2026-08-13_CBRS_Q2雲端業務
Cerebras Q2 快速推論雲端業務近 4 倍,產能擴增 > 10 倍
☘️ Article
孟恭觀點
- 這家爭取到滿多產能,後續就看和別人的機架結合,是否能交出公司答應的成效。
- Disaggregation 合作夥伴有 AMD Helios、AWS Trainium。
- OpenAI 貢獻顯著,隨 AWS、其他客戶 擴大,會稀釋佔比。
- HBM 架構在 吞吐量、速度 間做取捨,Cerebras SRAM 架構相反,支援極快速 token 生成,並維持中等程度吞吐量。
- 公司說今年產能比去年多 10 倍,明年又會多 3~4 倍。
- 以 AMD 合作為例,Helios 處理 prefill,Cerebras 做 decode。
- 與 AMD 的交易模式是自購自營:買 Helios 機架裝進自己的雲端,向客戶收費並承擔硬體 資本支出。
- AWS 合作要到 2027 年 Q1 才透過 Bedrock 正式上線,目前 254 億美元的 RPO 不包含 AWS/其他 Hyperscaler 合約。
- 公司觀察到新一代雲端業者正從依賴 Nvidia,轉向多供應商配置。
✍️ Abstract
Cerebras Q2 快速推論雲端業務近 4 倍
- 雲端業務近 4 倍:Cerebras Systems 2026 年 Q2 快速推論雲端業務接近 4 倍。
- 雲端營收成長:GAAP 雲端營收 年 +281%,核心雲端營收 年 +287%。
- 資料中心容量:目前已有 600 MW 容量簽約。
- 製造產能擴增:2026 年製造產能將擴增 > 10 倍。
- OpenAI 發布合作:成為 OpenAI 前沿模型 GPT-5.6 Sol 的發布合作夥伴。
- AMD、AWS 合作:兩項合作聚焦分散式推論。
孟恭觀點分析
- 產能擴張:今年產能較去年增加 10 倍,明年預期再增加 3~4 倍,後續取決於機架整合成效。
- 合作夥伴:Disaggregation 夥伴包含 AMD Helios、AWS Trainium。
- 客戶集中度:OpenAI 目前貢獻顯著,AWS、其他客戶 擴大後,OpenAI 佔比會稀釋。
- 架構取捨:HBM 在 吞吐量、速度 間取捨,Cerebras SRAM 支援快速 token 生成,吞吐量維持中等。
- 推論分工:AMD 合作由 Helios 處理 prefill,Cerebras 負責 decode。
- 自購自營:Cerebras 買入 Helios 機架並裝進自家雲端,直接向客戶收費,承擔硬體資本支出。
- AWS 上線:合作預計 2027 年 Q1 透過 Bedrock 上線,254 億美元 RPO 尚未包含 AWS/其他 hyperscaler 合約。
- 供應商分散:新一代雲端業者正從依賴 Nvidia,轉向多供應商配置。
專有名詞
- Disaggregation:將推論流程拆分為 prefill、decode 等階段的架構,合作夥伴包含 AMD Helios、AWS Trainium。
- OpenAI:目前對 Cerebras 雲端業務貢獻顯著的合作對象。
- HBM (高頻寬記憶體):需在 吞吐量、速度 之間取捨的記憶體架構。
- SRAM (靜態隨機存取記憶體):Cerebras 使用的記憶體架構,支援快速 token 生成。
- Prefill (預填充):模型處理輸入內容的階段,在 AMD 合作中由 Helios 處理。
- Decode (解碼):模型生成輸出的階段,在 AMD 合作中由 Cerebras 處理。
- RPO (剩餘履約義務):尚未認列的合約收入,目前金額為 254 億美元。
- Hyperscaler (超大規模雲端業者):AWS 等大型雲端基礎服務提供商。
